Micron Document
`:top
Der `!Universal Coded Character Set`! (kurz `!UCS`!, `F33f`_`[englisch`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Englische_Sprache]`_`f für `*Universeller codierter Zeichensatz`*) ist ein `F33f`_`[Zeichensatz`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Zeichensatz]`_`f, der in der internationalen `F33f`_`[Norm`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Normung]`_`f `!ISO/IEC 10646`! definiert ist. Seit der Revision 2011 (ISO/IEC 10646:2011) sind die definierten `F33f`_`[Zeichenkodierungen`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Zeichenkodierung]`_`f einschließlich ihrer Benennungen identisch mit denen des Unicode-Standards: `:cite-ref-0-1-0[`F5bf`_`[1`#cite-note-0-1]`_`f]

• `F33f`_`[UTF-8`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=UTF-8]`_`f
• `F33f`_`[UTF-16`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=UTF-16]`_`f
• `F33f`_`[UTF-32`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=UTF-32]`_`f

Ältere Ausgaben der Norm definierten andere Kodierungen, die jetzt `F33f`_`[deprecated`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Deprecated]`_`f sind:

• UCS-2, Untermenge von UTF-16
• UCS-4, als Kodierung identisch mit UTF-32

Der Unterschied zwischen UCS-2 und UTF-16 ist folgender:

• UCS-2 ist eine `F33f`_`[Fixed-Byte-Kodierung`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Double_Byte_Character_Set]`_`f: jedes Zeichen ist genau 2 Byte lang. UCS-2 kann damit die 65.536 Zeichen der `F33f`_`[Basic Multilingual Plane`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Basic_Multilingual_Plane]`_`f (BMP) darstellen.
• UTF-16 ist eine `F33f`_`[Flexible-Byte-Kodierung`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Multibyte_Character_Set]`_`f: ein einzelnes Zeichen ist 2 Byte oder 4 Byte lang – 2 Byte bei Zeichen in der oben genannten BMP, 4 Byte bei Zeichen außerhalb der BMP.

Dadurch hat jedes UCS2-Zeichen den gleichen `F33f`_`[Codepoint`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Codepoint]`_`f wie das entsprechende UTF-16-Zeichen, aber nicht jedes UTF-16-Zeichen kann in UCS-2 dargestellt werden (wenn es nämlich in UTF-16 vier Byte umfasst).

Der UCS wird entwickelt von `F33f`_`[ISO`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=International_Organization_for_Standardization]`_`f/`F33f`_`[IEC`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=International_Electrotechnical_Commission]`_`f/JTC1/SC2/WG2. Die Gruppe arbeitet sehr eng mit dem `F33f`_`[Unicode-Konsortium`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Unicode-Konsortium]`_`f zusammen, das die Standards ständig in neuen Versionen synchronisiert. Aufgrund dessen sind alle Kodierungen aus Gründen der `F33f`_`[Interoperabilität`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Interoperabilität]`_`f beschränkt auf die bei Unicode erlaubten 1.112.064 Zeichen (= 220+216, abzüglich 211 = 2048 Surrogate von UTF-16), nämlich von U+00000 bis U+0D7FF sowie von U+0E000 bis U+10FFFF.

Ursprünglich wurden diese beiden Formate definiert:

• UCS-2: `F33f`_`[obsolete`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Obsoleszenz]`_`f Kodierung in 2 `F33f`_`[Byte`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Byte]`_`f; dabei lässt sich nur die `F33f`_`[Basic Multilingual Plane`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Unicode]`_`f kodieren. Dies ermöglicht die Kodierung der meisten `F33f`_`[lebenden Sprachen`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Lebende_Sprache]`_`f und der gebräuchlicheren `F33f`_`[Sonderzeichen`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Sonderzeichen]`_`f. UCS-2 ist nicht mehr Bestandteil des Standards. UCS-2 war auch der `F33f`_`[Zeichensatz`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Zeichensatz]`_`f von `F33f`_`[Microsoft Windows NT`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Microsoft_Windows_NT]`_`f, wohingegen seit `F33f`_`[Windows 2000`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=Windows_2000]`_`f `F33f`_`[UTF-16`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=UTF-16]`_`f eingesetzt wird.
• UCS-4: Kodierung in 4 Byte (entspricht `F33f`_`[UTF-32`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=UTF-32]`_`f).

In der Version ISO/IEC 10646-3:2003 wurden die gleichen Formate `F33f`_`[UTF-8`:/page/entry.mu`zim=wikipedia_de_all_nopic_2026-01.zim|entry_path=UTF-8]`_`f, UTF-16 und UTF-32 beschrieben wie in Unicode 4.0.

>>Contents

• `F0af`_`[Gegenüberstellung der Versionen`#gegen-berstellung-der-versionen]`_`f
• `F0af`_`[Weblinks`#weblinks]`_`f
• `F0af`_`[Einzelnachweise`#einzelnachweise]`_`f

-─

>>Gegenüberstellung der Versionen

`:cite-ref-0-1-1[`F5bf`_`[1`#cite-note-0-1]`_`f]

• ISO/IEC 10646-1:1993 ≈ Unicode 1.1

• plus ISO/IEC 10646-1:1993/Amd 5:1998 bis ISO/IEC 10646-1:1993/Amd 7:1997 ≈ Unicode 2.0/2.1

• ISO/IEC 10646-1:2000 ≈ Unicode 3.0

• plus ISO/IEC 10646-2:2001 ≈ Unicode 3.1
• plus ISO/IEC 10646-1:2000/Amd 1:2002 ≈ Unicode 3.2

• ISO/IEC 10646-3:2003 ≈ Unicode 4.0

• plus ISO/IEC 10646:2003/Amd 1:2005 ≈ Unicode 4.1
• plus ISO/IEC 10646:2003/Amd 2:2006 ≈ Unicode 5.0
• plus ISO/IEC 10646:2003/Amd 3:2008 und ISO/IEC 10646:2003/Amd 4:2008 ≈ Unicode 5.1
• plus ISO/IEC 10646:2003/Amd 5:2008 und ISO/IEC 10646:2003/Amd 6:2009 ≈ Unicode 5.2

• ISO/IEC 10646:2011 ≈ Unicode 6.0
• ISO/IEC 10646:2012 ≈ Unicode 6.1/6.2/6.3

• plus ISO/IEC 10646:2012/Amd 1:2013 und ISO/IEC 10646:2012/Amd 1 ≈ Unicode 7.0

• ISO/IEC 10646:2014 und ISO/IEC 10646:2014/Amd 1:2015 ≈ Unicode 8.0

• plus ISO/IEC 10646:2014/Amd 2:2016 ≈ Unicode 9.0

• ISO/IEC 10646:2017 ≈ Unicode 10.0
• ISO/IEC 10646:2020 ≈ Unicode 13.0

• ISO/IEC 10646:2020/Amd 1:2023 ≈ Unicode 15.0

>>Weblinks

• `*Freely Available Standards`* mit ISO/IEC 10646 bei der ISO

>>Einzelnachweise

`:cite-note-0-1`!1.`! `F0af`_`[↑`#cite-ref-0-1-0]`_`f `*The Unicode® Standard Version 10.0 – Core Specification: Appendix C Relationship to ISO/IEC 10646.`* The Unicode Consortium, S. 907–908, abgerufen am 12. April 2018 (englisch).

`c`F0af`_`[↑ Back to top`#top]`_`f`a